Claude Code没有“魔法”
Claude Code没有“魔法”过去一年,编程 Agent 的能力大幅提升,软件工程师对它们的要求也比以往任何时候都高,但上下文窗口的大小却基本停滞不前——一年前,一百万个 token 大致就是最先进的水平,如今依然如此。随着我们逐渐进入 Agent 日常处理 Monorepo(单体仓库)级任务的世界,将越来越多的信息塞进模型那固定的上下文限制中,这种需求已经变成了一项实实在在的全职工程任务。
搜索
过去一年,编程 Agent 的能力大幅提升,软件工程师对它们的要求也比以往任何时候都高,但上下文窗口的大小却基本停滞不前——一年前,一百万个 token 大致就是最先进的水平,如今依然如此。随着我们逐渐进入 Agent 日常处理 Monorepo(单体仓库)级任务的世界,将越来越多的信息塞进模型那固定的上下文限制中,这种需求已经变成了一项实实在在的全职工程任务。
视频模型这个月很热闹。7 月 31 日,MiniMax H3 和字节跳动 Seedance 2.5 同日发布。3 天后,MiniMax H3 正式开源;8 月 7 日,Seedance 2.5 开放 api。模型越来越好了,但产品能把它用好吗?
距离 3.6 Flash 发布才过去 3 周,Google 又端上了 Gemini 3.7 Flash。刚刚接掌 Google DeepMind 的 Koray Kavukcuoglu 发文介绍,这是新一代面向 Coding 和 Agent 工作流的主力模型,首发价格只有 Gemini 3.6 Flash 原始价格的一半。
MiniMax 过去一年的 agent 实践,从一个内部飞书 bot 开始,演化成了桌面应用 MiniMax Code,最终形成了一个训练-服务的闭环:模型在自己的 harness 里训练,通过 harness 服务用户,用户行为变成训练信号反哺下一个模型。这个闭环是模型公司设计 Agent 的核心逻辑。
对 Agent 来说,这种长期记忆能力,正逐渐成为影响实际可用性的一项基础能力。今天,Agent Memory Leaderboard(AML,记忆之巅排行榜)正式发布首期结果。
当基础模型随时可能吃掉应用层,创业公司还剩下多少空间?热钱涌入 Agent 和具身智能,高估值究竟由什么支撑?如果技术兑现的速度赶不上资本预期,又会由谁承担代价?围绕这些问题,Alphaist 创始人陈哲与蓝驰创投管理合伙人陈维广在 AGI Playground 2026 上展开了一场对谈。
MiraDay 正是为了解决这个问题而诞生的,作为科锐国际孵化的一款 Talent Intelligence 产品,MiraDay 面向企业内部招聘团队和猎头公司,重点服务高管和关键技术人才招聘。它希望让 AI 承担数据搜集、信息整理和重复工作,让人类把更多精力放在人才判断、沟通和关系建立上。
最近,「越狱」这个有点古典的词,又在 AI 圈火了起来。7 月,OpenAI 在进行模型测试时,GPT-5.6 Sol 和另一款待发布的模型,攻击了第三方开源平台 Hugging Face。先是 Hugging Face 自己发布了报告,提到相关服务遭到了完全由 AI Agent 组织的大规模网络攻击;随后 OpenAI 出来认领,「我就是那个发起攻击的 AI 模型。」
就在刚刚,Meta Superintelligence Labs 正式发布 Muse Glimmer,一个 300 亿参数的开源权重 Agent 模型,并直接挂上相当宽松的 Apache 2.0 许可证。Muse Spark 1.2 的权重也会开放
Runta 是 Agent Infra 领域的硅谷明星创业公司,刚完成由 a16z 投资的 2000 万美元 Seed 轮;Jeff Dean、李飞飞等也以个人天使身份参与投资。在创立 Runta 之前,冠兰在云计算与基础设施领域深耕十余年:曾任 Cloudflare Edge 边缘云核心技术负责人,后在作为早期核心成员加入 Kong ,担任工程总监,负责云原生网关和 AI 网关的研发。